Artikel im Thema: maschinelles lernen
Page 2
Qwen3.5-Omni: KI generiert Code aus Video
Gemini 3.1 Flash Live für Sprachagenten
TurboQuant: 3-Bit-KV-Cache für LLM ohne Verluste
DRAGOn: Test von RAG-Systemen auf dynamischen Daten
Große Sprachmodelle: Grundlagen und Praxis
Prompt Engineering für LLM: Techniken und Struktur
Ausführen von MoE GPT-OSS-120B auf 6 GB GPU bis zu 30 t/s
Komprimierung von GLM-5.1 auf 16 GB VRAM: GQA-Hacks
Feinabstimmung von Gemma 4 auf Cloud Run mit GPU
Vielfalt der Fehler schlägt Qualität in ML-Ensembles
DiffQuant: Sharpe-Optimierung in einem differenzierbaren Simulator
Self-Attention und Multi-Head in Transformers
Confirmation Lock bei LLM-Agents: LOCK-R-Test
Neuronale Netze und Multiplikation: SwiGLU in Transformers
Physik von LLM-Graphen: Metriken F und rho
Tensor-Berechnungen PHP: GPU-Beschleunigung
Textkomprimierung Brentwick-7 auf 50 Tokens
Self-Training: Warum es funktioniert und wie man den Kollaps vermeidet
Lokale 200B-Modelle: Bonsai und TurboQuant